WeChat Vision Team Opensources General Multimodal Embedding Model WeMM-Embedding, Daily Call Volume Exceeds Ten Billion
Tencent WeChat Vision Team open-sourced WeMM-Embedding, a multimodal embedding model supporting text and image inputs. It offers 2B, 4B, and 9B versions for different deployment needs, with a unified architecture and training strategy, aiming to support AI developers and drive vertical innovations.....